AI资讯新闻榜单内容搜索-Agent

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Agent
全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?

全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?

全网最硬核 OpenClaw 2.0 实测:从 ToC 到 ToB 的试探,Agent 网关能重塑工作流边界吗?

OpenClaw 2.0(v2026.8.1)对比前代v2026.7.1-2的实测显示,新版将LLM请求次数减少38%、工具调用减少35%且未触发上下文压缩,把开源Agent从个人工具推向可长期托管、可协作复盘的工作系统,但命令行安装和工程门槛依然较高,更适合团队受控环境测试。

来自主题: AI产品测评
8993 点击    2026-09-05 11:08
装上Superdesign,立刻让 Codex 变成设计专家

装上Superdesign,立刻让 Codex 变成设计专家

装上Superdesign,立刻让 Codex 变成设计专家

Superdesign 近日在 Codex(ChatGPT)插件市场上线官方插件,可让 Codex 自动扫描项目设计资产并在右侧画布流式渲染 UI,Agent 还会自检迭代,用户选定后一键将设计代码应用回本地项目。

来自主题: AI资讯
9093 点击    2026-09-05 10:53
腾讯、字节、阿里「会战」AI 办公之后:Agent 领域格局已变

腾讯、字节、阿里「会战」AI 办公之后:Agent 领域格局已变

腾讯、字节、阿里「会战」AI 办公之后:Agent 领域格局已变

创新工场汪华与Floatboat.ai创始人谭少卿对话指出,腾讯WorkBuddy、字节豆包工作、阿里千问办公等大厂AI办公会战已完成Agent市场教育,GLM-5.3-Flash和DeepSeek-V4-Flash等国产模型跨过能力门槛,巨头的壁垒仅剩资金,而中国创业者凭借贴近开源模型生态的优势,有望在垂直Agent领域找到更多机会。

来自主题: AI资讯
6144 点击    2026-09-05 10:46
RSI离我们有多远?这家中国团队给出了第一梯队的工程解

RSI离我们有多远?这家中国团队给出了第一梯队的工程解

RSI离我们有多远?这家中国团队给出了第一梯队的工程解

Agent 经常遇到这样一种幻觉:你给模型接入了终端,下发了一个复杂的 debug 任务,看着它顺藤摸瓜排查了几个小时,最终完美修复了依赖冲突,甚至连测试用例都帮你补齐了。

来自主题: AI技术研报
8885 点击    2026-09-03 14:17
Agent正确率从26%飙到70%,最近爆火的EvoX有东西啊

Agent正确率从26%飙到70%,最近爆火的EvoX有东西啊

Agent正确率从26%飙到70%,最近爆火的EvoX有东西啊

Agent 出现这么久了,大伙应该对它们的工作方式也不陌生了吧?

来自主题: AI资讯
7547 点击    2026-09-02 15:02
33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。

来自主题: AI技术研报
8085 点击    2026-09-02 14:33
苹果被骂惨的设计,在 AI 时代迎来高光时刻

苹果被骂惨的设计,在 AI 时代迎来高光时刻

苹果被骂惨的设计,在 AI 时代迎来高光时刻

已经被苹果打入冷宫三年的 Touch Bar,最近意外迎来事业上的「第二春」。

来自主题: AI资讯
10046 点击    2026-09-02 10:04
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

图片不只被编码,还直接参与 Attention、MoE 与 Agent 推理。

来自主题: AI技术研报
9823 点击    2026-09-02 09:27
刚刚,Claude 5.1 发布!全球最强模型来了

刚刚,Claude 5.1 发布!全球最强模型来了

刚刚,Claude 5.1 发布!全球最强模型来了

Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,Fable 5.1 多项基准测试超越上一代,缓存读取成本降低 75%,典型任务整体费用降低约 25%、高 Agent 化任务最高降低约 45%,Mythos 5.1 则面向经审核的高风险领域合作伙伴提供更宽松能力并采用更严格的访问控制。

来自主题: AI资讯
9704 点击    2026-09-02 08:50
谷歌重磅发布WikiSkill,技能可以自己进化了!

谷歌重磅发布WikiSkill,技能可以自己进化了!

谷歌重磅发布WikiSkill,技能可以自己进化了!

一个 Agent 到底凭什么越来越强?有人靠更大的模型,有人靠更多数据。就在前天,Google Research 最新发布的 WikiSkill 给出了另一条答案:给 Agent 搭一套三层知识架构,让技能自己进化。

来自主题: AI技术研报
7002 点击    2026-09-01 10:27